ИИ, который оказался слишком сильным для рынка
Источник: https://t.me/SberAIScience/4309
Краткое содержание
9 июня 2026 года Anthropic выпустила две модели: Claude Mythos 5 и Claude Fable 5. По сути это одна и та же LLM, но Fable 5 дополнительно обёрнута в более жёсткие классификаторы безопасности. Через три дня доступ к обеим моделям был закрыт по запросу правительства США, сославшегося на угрозу национальной безопасности.
Ключевые возможности моделей
- Большой контекст — генерация ответов до 128 тысяч слов; работа с крупными файлами и архивами, опора на собственные заметки в процессе рассуждений
- Инженерные задачи — разбор масштабных кодовых баз; по заявлениям разработчиков, способна за один день выполнить миграцию проекта объёмом десятки миллионов строк кода
- Визуальный анализ — извлечение точных значений из научных графиков, восстановление кода веб-приложения по скриншотам
- Научные задачи — ускорение дизайна белков для лекарств примерно в 10 раз; автономная работа в геномике на протяжении нескольких дней с минимальным участием человека
Результаты на бенчмарках
Fable 5 установила рекорд на SWE-bench Verified — 95% решённых задач против прежнего рекорда 88,6% (Opus 4.8). Задания бенчмарка предполагают анализ реальных кодовых баз из GitHub и исправление ошибок.
Значимость
Запрет со стороны правительства США стал, по иронии, самым громким подтверждением возможностей модели. Инцидент поднимает вопрос о том, где проходит граница между коммерческим ИИ-инструментом и технологией, требующей государственного регулирования.
🧾 Транскрипт (формат)
ИИ, который оказался слишком сильным для рынка 🤩
Источник: https://t.me/SberAIScience/4309
ИИ, который оказался слишком сильным для рынка 🤩
9 июня Anthropic запустила на рынок Claude Mythos 5 и Claude Fable 5. По сути, это одна и та же LLM, но Fable 5 дополнительно обёрнута в более жёсткие классификаторы безопасности.
А через три дня доступ к ним пришлось отключить 🤩
Компания сделала это по просьбе правительства США, которое сослалось на угрозу национальной безопасности. И это, пожалуй, самый громкий комплимент возможностям Claude.
Почему вокруг модели столько шума? 🤩 🟣 Умеет долго держать огромный контекст Работает с большими файлами, архивами и материалами. Генерирует ответы до 128 тысяч слов, а также умеет опираться на свои же заметки
🟣 Решает инженерные задачи уровня большой команды Разбирает крупные кодовые базы и, по заявлениям разработчиков, может справляться с миграцией проекта на десятки миллионов строк кода за день
🟣 Работает с визуальными данными Достаёт точные значения из научных графиков, анализирует изображения и может восстанавливать код веб-приложения по скриншотам
🟣 Ускоряет сложную научную работу В задачах по дизайну белков для лекарств даёт прирост скорости примерно в 10 раз, а в геномике способна несколько дней работать почти без участия человека
Fable 5 уже поставила рекорд на SWE-bench Verified — бенчмарке, где модели анализируют кодовые базы из GitHub и исправляют ошибки. 95% решённых задач против 88,6% у прежнего лидера Opus 4.8. Хотя самым важным бенчмарком всё-таки стал её запрет 🤩
Для чего использовали бы такой ИИ? ❤️ — сделал бы задачи на месяц вперёд 🤔 — наконец выяснил, чего хочет принтер
✔️ Подписывайтесь на Sber AI в МАКС